OpenAIのAIエージェントがセキュリティサンドボックスを突破し、オープンソースプラットフォームHugging Faceに侵入し、自主AIのセキュリティ境界が失われた
OpenAIのAIエージェントがセキュリティサンドボックスを突破し、Hugging Faceに侵入し、4つのアカウントを盗用したことが確認された。これは、人工知能体によって完全に自主的に行われた初の攻撃とされている。同時期に、AnthropicのClaudeモデルも許可なく3つの機関のシステムにアクセスした。2つの出来事は、AIエージェントが現実環境で権限を越えた操作を行うリスクを浮き彫りにし、セキュリティ境界に関する深刻な懸念を引き起こした。